De fotos, capturas de tela e PDFs digitalizados, Imagem para textoe o OCR de PDF são processados diretamente no seu dispositivo. Páginas PDF com texto selecionável são lidas da camada de texto em vez de usar OCR.
JPG, PNG, WebP, BMP, PDF · Os arquivos originais não são enviados ao servidor da MISCLAND.
Não. As imagens e os PDFs originais selecionados não são enviados ao servidor; eles são processados na memória do navegador atual.
Os cálculos de OCR são executados no seu PC ou dispositivo móvel usando PaddleOCR.js e WebAssembly. O servidor da MISCLAND apenas entrega arquivos estáticos do mecanismo OCR e dos modelos; ele não recebe nem armazena o conteúdo dos documentos ou os resultados do OCR.
Se uma página PDF já contiver texto selecionável, o PDF.js extrai esse texto diretamente. Esse método é mais rápido que OCR e preserva o texto original com maior precisão.
Somente páginas digitalizadas ou PDFs em formato de imagem sem camada de texto são renderizados como imagens no navegador e depois processados por OCR. Se um PDF misturar páginas com texto e páginas digitalizadas, cada página será tratada automaticamente pelo método adequado.
Você pode selecionar coreano, inglês, espanhol, português, francês, alemão, italiano, indonésio, vietnamita, árabe, hindi, chinês simplificado ou tradicional e japonês.
A ferramenta usa um modelo móvel de reconhecimento PP-OCRv5 adequado ao idioma selecionado. O modelo só é carregado quando você escolhe o idioma e inicia de fato o OCR, e o cache do navegador é usado nas execuções seguintes.
O OCR não pode garantir 100% de precisão, pois o reconhecimento varia conforme a qualidade da origem, o tamanho do texto, a inclinação, o fundo e a fonte.
Documentos impressos e digitalizações nítidas oferecem os melhores resultados. Use Alta qualidade para textos muito pequenos e experimente Aprimoramento do documento em digitalizações fracas em preto e branco. Sempre compare resultados importantes com o documento original.
Sim. Funciona em navegadores móveis modernos compatíveis com WebAssembly e Web Workers.
O OCR usa a memória e o poder de processamento do seu dispositivo, portanto aparelhos modestos ou documentos muito grandes podem demorar mais. Em dispositivos móveis, limites de segurança menores são aplicados automaticamente à quantidade de arquivos, tamanho total, páginas PDF e resolução das imagens.